技術2026年3月31日(火)約6分OllamaがMLXバックエンドに移行、Apple Siliconでのローカル推論が劇的に高速化Ollama 0.19がApple SiliconでのバックエンドをMLXに切り替え、プリフィル1810トークン/秒・デコード112トークン/秒を達成。NVFP4量子化サポートとキャッシュ改善も同時投入された。OllamaMLXApple SiliconLLMローカルLLM推論最適化
技術2026年3月26日(木)約10分ComfyUIアプデ後にQwen Image Editが10分かかるようになった原因を特定したMPSのBF16演算がFP16の2倍遅い問題と、FP16 Attentionバグが重なって発生した速度劣化の原因と対策ComfyUIQwenApple SiliconMPSPyTorch実験
技術2026年3月25日(水)約18分HypuraのNVMeストリーミングとTurboQuantのKVキャッシュ量子化llama.cppのmmap設計を脱却してNVMe 3層配置でDenseモデルもストリーミングするHypuraと、極座標変換で量子化定数オーバーヘッドを排除するTurboQuant。Flash-MoEとの設計比較、KVキャッシュ圧縮が実際に効くシナリオの整理も。LLMローカルLLM量子化Apple Silicon推論最適化KVキャッシュRust
技術2026年3月1日(日)更新約13分LTX-2とWan 2.2をM1 Max 64GBで動かせるのか調べて動かしたLTX-2とWan 2.2をM1 Max 64GBで動かした。FP8はMetal非対応、GGUF形式で回避。Wan 2.2は2秒に82分。LTX-2は公式パイプラインがMPSでNaNを出し、KSampler代替でも品質が実用に達しない。AI動画生成LTX-2WanApple Silicon実験
技術2026年2月13日(金)更新約5分ComfyUIのUpscaleがMac MPSで壊れる問題をcontiguousで直したLoad Image経由のUpscaleで画像が崩壊する問題を、テンソルのnon-contiguous対策で修正した記録。2026-04-29にComfyUI更新で上書きされて再発したのでPyTorch側の上流issueと再発の経緯も追記。ComfyUIApple SiliconPyTorchMPS実験
技術2026年2月3日(火)約4分M1 Max 64GBでQwen Image Edit(NSFW版)をローカル実行するApple Silicon MacでQwen-Rapid-AIO-NSFW v16を動かし、キャラ維持しながらポーズ変更する方法ComfyUIQwenApple Silicon画像生成実験
技術2026年2月3日(火)約4分NovelAI精密参照をローカルで再現する方法を調べた — ComfyUI + IP-AdapterNovelAIの精密参照(キャラ参照+絵柄参照)をComfyUI + IP-Adapterでローカル再現するための下調べ。セットアップ手順とパラメータ設定をまとめた。AI画像生成ComfyUIIP-AdapterNovelAIApple Silicon
技術2026年2月3日(火)約3分BEYOND_REALITY_Z_IMAGE — Z-Image Turboベースのフォトリアル人物特化モデルModelScopeで公開されているZ-Image Turboの派生チェックポイント。肌のテクスチャとフィルム写真的な美学に特化。M1 Max 64GBでも動作可能。画像生成AIZ-ImageApple SiliconComfyUI
技術2026年2月3日(火)約3分ACE-Step:ローカルで動く音楽生成AI基盤モデルを調べた音楽版Stable Diffusionを目指すACE-Stepについて、M1 Maxで試す前の下調べとしてまとめた。アーキテクチャ、機能、インストール手順など。AI音楽生成Apple SiliconMacPythonローカルAI
技術2026年2月3日(火)約3分Z-Image-Distilled — 蒸留で高速化しても多様性を維持したZ-Image派生モデルZ-Imageを蒸留で高速化したZ-Image-Distilledの概要。FLUX.1 Schnellとの違い、M1 Max 64GBでの動作、LoRA互換性についてまとめた。AI画像生成Z-ImageApple SiliconLoRA
技術2026年2月3日(火)更新約3分FLUX.2 Klein — 9Bパラメータの軽量画像生成モデルとApple Silicon対応状況Black Forest LabsのFLUX.2 Klein 9Bモデルの概要と、M1/M2/M3/M4 Macでの動作についてまとめた。メモリ帯域幅やFP8量子化など、CUDA vs MPSの性能差の要因も解説。AI画像生成FLUXApple SiliconMac
技術2025年12月9日(火)約7分【RAG】Mac mini M4 Pro + Difyで社内ヘルプデスクを構築する2025(前編)Mac mini M4 ProとDifyを使った社内ヘルプデスクRAGシステムの構築計画。2025年版Difyの進化ポイントと、ローカルLLM運用のコツをまとめました。AILLMRAGDifyMacApple SiliconOllamaDocker